Artykuły w temacie: uczenie maszynowe
Page 2
Meta-Harness optymalizuje LLM lepiej niż inżynierowie
Microsoft modele MAI: WER 3,8% i plany do 2027
Gemma 4: otwarte modele MoE Google do 31B parametrów
Qwen3.6-Plus: programowanie agentowe i multimodalność
Qwen3.5-Omni: AI generuje kod z wideo
Gemini 3.1 Flash Live dla agentów głosowych
TurboQuant: 3-bitowy KV-cache dla LLM bez strat
DRAGOn: test systemów RAG na danych dynamicznych
Duże modele językowe: podstawy i praktyka
Inżynieria promptów dla LLM: techniki i struktura
Uruchomienie MoE GPT-OSS-120B na 6 GB GPU do 30 t/s
Kompresja GLM-5.1 na 16 GB VRAM: hacki GQA
Dostrojenie Gemma 4 na Cloud Run z GPU
Różnorodność błędów pokonuje jakość w ansamblach ML
DiffQuant: optymalizacja Sharpa w różniczkowalnym symulatorze
Self-attention i multi-head w transformerach
Augmentacja bbox w Albumentations: formaty i błędy
Induction Heads na TinyStories: słabe formowanie
Confirmation Lock w agentach LLM: test LOCK-R